返回Gemma 4 31B

Gemma 4 31B

英伟达
2026-08-25 12:37:13

英伟达称 Groq 3 LPX 已全面投产,Gemma 4 31B 推理达 3400 token/秒

英伟达宣布 Groq 3 LPX 推理芯片已进入全面生产阶段,并称其在 Gemma 4 31B 模型上的推理速度达到每秒 3400 token。按英伟达说法,这一速度比 Cerebras 快 4 倍。不过报道同时提到,这一对比并不简单:英伟达至少需要 64 个加速器才能达到该速度,而 Cerebras 仅需 1 至 2 个。该架构在大型 MoE 模型上的扩展能力仍有待观察。

10
英伟达称 Groq 3 LPX 已全面投产,Gemma 4 31B 推理达 3400 token/秒
英伟达
2026-08-25 02:02:15

英伟达首测 Vera Rubin NVL72:DeepSeek Agent 任务吞吐最高增 30 倍

英伟达首次公布 Vera Rubin NVL72 片上实测数据,并以 DeepSeek-V4-Pro 运行 AgentX 智能体编码负载。官方数据显示,相比 GB300 NVL72,该系统每兆瓦吞吐量最高提升 30 倍、每百万 Token 成本最高下降 35 倍。英伟达同日还披露 Groq 3 LPX 已全面量产,Gemma 4 31B 在 10 万 Token 上下文窗口下输出速度达 3400 Token/秒,Vera CPU 也已进入部署阶段。

70
英伟达首测 Vera Rubin NVL72:DeepSeek Agent 任务吞吐最高增 30 倍
AI算力
2026-08-18 08:13:29

台湾数位产业署免费 AI 算力申请进入最后梯次

台湾数位发展部数位产业署 115 年度免费 AI 算力平台申请已进入后段,全年收件将于 10 月 30 日截止。符合资格的国内业者经核定后,可免费使用 3 个月 GPU 算力,用于训练、微调开源模型,或通过 API 串接预装大语言模型。官方称,截至 114 年底,已有 186 家 AI 新创与资服业者使用平台,产出至少 266 个模型或创新应用。

660
台湾数位产业署免费 AI 算力申请进入最后梯次